扫描下载APP
其它方式登录
文章探讨AI行业从早期狂热拉拢普通用户(C端)转向聚焦企业客户(B端)的战略转变,以豆包、千问、百度、DeepSeek等为例,指出2亿日活的普通用户因变现能力弱而被边缘化,大厂转向产业智能体、办公机器人等商业化路径,强调普通用户虽暂非收入主力,但其数据和交互仍是大模型迭代不可或缺的基础资源。
OpenAI推出GPT-6 Sol和Luna两款新模型,以能力下放、价格腰斩(降幅50%)策略直击DeepSeek等竞品,主打高性价比AI服务;两者均支持百万级上下文、多模态输入及可调推理强度,在代码审查、Agent任务等场景表现接近旗舰模型但成本大幅降低。
DeepSeek公开31页系统论文,首次披露其自研沙箱平台DSec,该平台支撑V3.2至V4.1全部Agentic RL训练,日均服务300万个沙箱、峰值并发超38万,具备高密度调度、分层镜像加载与安全防护能力,标志着Agent训练竞争从算法层转向环境基建层。
DeepSeek联合清华大学发布DSec沙盒基础设施,用于大规模Agent训练,通过可组合层、按需加载镜像和资源精算三大机制提升效率;论文第6节隐含RSI(递归自我改进)雏形,即Agent自主构建训练环境形成闭环,标志着AI基础设施竞争正从模型能力转向安全、高效的执行环境。
兆易创新创始人朱一明通过其关联产业资本石溪资本,拟出资50亿元参与AI公司DeepSeek第二轮融资,凸显产业资本深度介入AI与半导体融合趋势;石溪资本依托兆易创新、长鑫科技等半导体资源,专注硬科技投资并密集收获科创板IPO,体现产业资本在技术赋能与生态协同上的核心优势。
小米MiMo大模型团队负责人罗福莉提前披露MiMo-V3核心架构HySparse2,该架构通过两级KV共享和Token级稀疏选择,显著降低长上下文下的Prefill计算量(降至Hybrid SWA的约1/5)和KV Cache占用(降至约1/4.5),并提升Agent多轮任务中的长上下文检索准确率。
DeepSeek创始人梁文锋署名的新论文公开了其自研Agent训练沙盒平台DSec(DeepSeek Elastic Compute)的技术细节,该平台支持大规模、高并发的Agent强化学习训练,具备单日300万个沙盒服务能力、多后端环境统一调度、分层镜像按需加载及安全隔离等能力,解决了Agent训练中环境规模化、资源高效利用与执行风险控制等核心难题。
DeepSeek正在进行严格筛选的第二轮融资,计划募资500亿元、估值5000亿元,已吸引大量LP激烈抢筹,但因严控LP资质(如剔除国资、非上市公司及自然人等)导致进度延迟;融资或超募,且与科创板上市计划紧密关联,目标2027年挂牌。
文章以DeepSeek两位关键人物——应届毕业即负责核心算子的刘胜与和环境科班出身、无财务经验的新任CFO严文韬——为切入点,剖析其独特管理逻辑:重好奇心与能力而非资历,强调自下而上分工、扁平化授权;在快速扩张与筹备科创板上市背景下,CFO角色被重新定义为服务资本估值、团队稳定与长期研发投入的枢纽,反映AI公司治理从初创灵活向制度化演进的张力。
DeepSeek发布新论文,公开其Agent训练基础设施DSec系统,该系统通过四种隔离后端(FnCall、Container、MicroVM、Full VM)支持多样化Agent任务,实现每秒5000+沙盒的高密度调度与按需加载,同时应对Agent作弊、内核崩溃等安全挑战,强调Agent训练对环境构建、资源调度和安全围栏的全新工程要求。
OpenAI发布GPT-6 Sol和Luna新模型,API价格大幅下调至前代约一半,Luna单价已逼近DeepSeek V4.1 Flash的普通请求价格,直接挑战其低价优势;同时通过缓存优化、推理强度分级和产品矩阵(Codex/Work/API)强化成本效益,推动大模型竞争从性能比拼转向单位任务成本与规模化效率之争。
DeepSeek宣布将模型参数规模推进至8万亿,加入国内大模型厂商新一轮超大参数竞赛;月之暗面Kimi K3、字节、阿里等头部机构亦纷纷布局5万亿至10万亿参数模型,背后驱动力是MoE架构普及与Agent时代对模型能力覆盖面和长任务稳定性的更高要求。
朱啸虎因坚持商业化验证逻辑,早期看空并回避国内基础大模型创业,错失智谱、MiniMax、DeepSeek、月之暗面等公司高速成长与上市红利;虽后期认可DeepSeek技术突破,但因估值过高未参与其510亿元A轮融资,凸显其移动互联网时代投资方法论在AI硬科技长周期、高投入赛道中的适配困境。
90后前高瓴创投合伙人严文韬正式加入AI公司DeepSeek担任CFO,终结其成立三年来的CFO空缺;此举正值DeepSeek临近二轮融资关键期,融资估值升至5000亿元,并启动严格LP筛选,同时筹备科创板IPO,市场对其估值预期已达万亿元。
文章讲述幻方(DeepSeek)与华为在中美科技封锁背景下被迫深度协同的故事:幻方创始人梁文锋以超前算力储备应对英伟达禁令,DeepSeek通过极致工程优化在阉割芯片上训练出高性能大模型;华为昇腾芯片则借DeepSeek模型实现生态验证。双方最终联合推进16万颗昇腾芯片的国产算力底座建设,将技术突围押注于内蒙古绿电草原,体现‘必须成功’的生存级战略绑定。